從照片、截圖與掃描 PDF 中,圖片轉文字與 PDF OCR 都直接在你的裝置上處理。含可選取文字的 PDF 頁面會直接讀取文字層,而不是執行 OCR。
JPG、PNG、WebP、BMP、PDF · 原始檔案不會上傳到 MISCLAND 伺服器。
不會。您選擇的原始圖片與 PDF 不會上傳到伺服器,而是在目前瀏覽器的記憶體中處理。
OCR 計算透過 PaddleOCR.js 與 WebAssembly 在您的 PC 或行動裝置上執行。MISCLAND 伺服器只提供靜態 OCR 引擎與模型檔案,不會接收或儲存文件內容或 OCR 結果。
如果 PDF 頁面本身已有可選取文字,PDF.js 會直接擷取。這比 OCR 更快,也能更準確地保留原始文字。
只有沒有文字層的掃描頁面或圖片型 PDF 才會在瀏覽器中轉成圖片後進行 OCR。若同一份 PDF 同時包含文字頁面與掃描頁面,系統會逐頁自動選擇適合的處理方式。
可選擇韓文、英文、西班牙文、葡萄牙文、法文、德文、義大利文、印尼文、越南文、阿拉伯文、印地文、簡體或繁體中文以及日文。
本工具會使用適合所選語言的 PP-OCRv5 行動版辨識模型。只有在選擇語言並實際開始 OCR 時才會載入該模型,之後使用會利用瀏覽器快取。
OCR 無法保證 100% 準確,因為辨識結果會受原始品質、字體大小、傾斜、背景與字型影響。
清晰的印刷文件與掃描件效果最佳。文字很小時請使用高品質模式;較淡的黑白掃描件可嘗試文件增強。重要內容請務必與原始文件核對。
可以。支援 WebAssembly 與 Web Worker 的現代行動瀏覽器皆可使用。
OCR 會使用您裝置的記憶體與運算資源,因此低階裝置或非常大的文件可能需要較長時間。在行動裝置上,系統會自動對檔案數量、總大小、PDF 頁數與圖片解析度套用較低的安全上限。